雷峰网
09-04 07:00
拆解 Claude 5.1:38 小时不睡觉的背后,Anthropic 正在终结「模型论」
📌 一句话:Anthropic用38小时持续任务能力证明,AI竞赛已从“参数大小”转向“真实可用”,只会跑分的模型正在被淘汰。
💡 3个要点
长程任务突破:Claude 5.1能稳定运行38小时处理复杂任务,这意味着AI终于能从“问答玩具”变成真正的“工作助手”
重新定义竞争维度:Anthropic不再堆参数,而是死磕“任务完成率”,逼迫整个行业放弃PPT式宣传
用户用脚投票:当AI能真正帮人完成任务而不是制造更多问题时,参数排名将变得毫无意义
📖 背景
大模型军备竞赛持续升温,各家都在吹嘘参数规模和benchmark分数,但用户真正需要的——长时间稳定完成任务——始终是痛点。Anthropic选择在这个节点秀出“续航”肌肉,显然是有备而来。
💭 点评
“模型论”的终结是迟早的事。当行业集体陷入参数焦虑时,Anthropic这步棋走得很聪明:不再教你AI有多强,而是直接展示它能陪你“加班”到天亮。这不只是在秀技术,更是在改变评价AI的逻辑——从“我能做什么”变成“我能为你做什么”。国内厂商该醒醒了,堆参数的玩法快玩不下去了。
📖 原文链接
点击阅读原文 →